英伟达有点危险了，因为 DeepSeek 要出新的模型了。你还记得去年 DeepSeek 出新模型的时候，英伟达有多惨吗？今年大家说，好像没有去年那么爆炸，但是英伟达处的社会地位也不一样了呀。它现在也是前有狼、后有虎。

怎么讲？因为之前英伟达是推理、训练两条腿走路，都得用它家的东西。但是现在推理侧，因为云服务商的出现，已经不那么依赖于它的显卡了。为什么？因为云服务商直接就把 CUDA 这个事情给绕开了。上一次我跟大家说绕开的时候，大家说不信是吧？现在是实实在在的，在推理侧，CUDA 没那么重要了。

你不管有什么样的模型，往上一提，接口一接，然后你说你去找 GPT，那你就去找 GPT；你说你去找 Kimi，去找 MiniMax，都没问题。剩下的就压根不用你管，你知道吗？更不用说它后边这个硬件到底是英伟达还是昇腾，根本不用你管。

那现在就变成两条路了。第一条路，我直接走国产的模型，比如说我用的是 Kimi，背后用的是英伟达卡也好，昇腾卡也好，最后在中国的供电系统下把这个东西算完，它便宜不便宜？那当然便宜了。我们的成本，连模型、算力、电力全加在一起，也就是美国那边的十分之一。

那你十分之一，在前一段时间大家发酵那个什么 OpenCloud、那个“龙虾”是吧，大量用 agent 消耗算力的情况下，美国人也花不起呀。所以在推理侧，就是春节期间，大家知道有两个我们港股上市的公司涨得非常猛。为什么？因为大家在用 agent 的时候发现，哎呀，国外的太贵了，外国人都跑到中国来用这个模型了。所以推理侧现在英伟达并不是那么占优。

那还好，所有的这种，不管你是 Kimi 也好，还是 GPT 也好，大部分现在训练其实还得用英伟达的卡。你别管禁令不禁令，是吧，我偷偷用也得用。毕竟训练得用大规模的卡做底层，然后不容得一丝差错，是吧，大部分还是在用英伟达、CUDA 去练。

但是最近一个消息，新出来的这个 V4 模型，我不准备先去给英伟达和 AMD 做优化了。那什么意思啊？这就引人遐想了。有两种可能。第一种可能说，你还是用英伟达的卡训练的，但是为了让国产厂商能够跟英伟达站在一样的起跑线上，是吧，我也给昇腾去做一些适配。

但还有一种可能，就是压根我训练就没用英伟达。为什么呢？毕竟 DeepSeek 是全球瞩目的一款模型，每次出来之后，它都是以小而美著称的。而这个小而美，如果再配上用国产算力去做训练，那它真的又要炸一次了。

它这个炸在两个方面。第一个方面，你训练如果都不用英伟达了，那英伟达是不是另一条腿立马又给打折了？然后大家说，那没问题，美国那些人还在用英伟达呢。美国人现在喜欢用英伟达吗？你去看一看 Gemini，是不是自己用自己的芯片在做训练？它用一部分 TPU，用一部分英伟达，大部分还是用它自己的吧。

然后你再去看大模型 Grok，马斯克自己也在想着去建芯片。然后你再去看 OpenAI，之前跟英伟达应该签了 1000 亿的合同，现在缩减到 300 亿了，分批。这一系列的一系列指向的就是：英伟达现在是前有狼、后有虎，就等着能不能给出一记暴击来了。我们拭目以待。
